2026 09 06 Astra 최근 논의와 대비 전략

📅 2026-09-06 11:10 · obsidian-share

title: Astra 최근 논의와 대비 전략

type: note

status: summarized

source_type: research-synthesis

knowledge-candidate: true

created: 2026-09-06

updated: 2026-09-06

topics:

- GPT-6 Astra

- AI agents

- AGENTS.md

- Skills

- Prompt engineering

- Codex

keywords:

- instruction following

- progressive disclosure

- reasoning effort

- completion criteria

- human approval boundary

source:

- https://x.com/gencoin8/status/2096107750589857989?s=46

- https://developers.openai.com/api/docs/guides/latest-model


Astra 최근 논의와 대비 전략

한 줄 요약

Astra 전환의 핵심은 스킬을 전부 지우는 것이 아니라, 예전 모델의 부족함을 보완하려고 쌓은 중복·과잉 지시를 줄이고, 중요한 지식·안전 경계·완료 기준만 선명하게 남기는 것이다.[2][3][4]

이번 조사의 결론

  • 공유된 X 글의 핵심 방향은 맞다. OpenAI의 Victor E. Nunez는 Astra rollout을 계기로 AGENTS.md, Skills, reasoning level을 다시 점검하라고 말했다.[1][2]
  • 다만 이것은 “OpenAI의 긴급 공지”라기보다 OpenAI 관계자의 실무 권고에 가깝다. “모든 스킬이 무용해졌다”거나 “코딩 스킬은 확실히 해롭다”는 해석은 원문과 공식 문서가 직접 뒷받침하지 않는다.[1][2][6]
  • OpenAI 공식 문서는 Astra가 이전 모델보다 지시를 더 강하게 따르고, Skills와 AGENTS.md 안의 지시에 더 민감할 수 있으므로 해당 파일을 감사하라고 명시한다.[4]
  • 디오의 현재 환경에서는 기존 지침을 당장 대량 삭제할 필요가 없다. 프로젝트별 AGENTS.md는 비교적 짧고 브랜드·독자·발행 규칙처럼 모델이 대신 알 수 없는 고유 정보를 담고 있으며, 전역 ~/.codex/AGENTS.md는 비어 있었다.
  • 지금 필요한 것은 삭제 작업이 아니라 Astra 전환 전 감사 → 작은 실험 → 필요한 것만 수정이다.
  • 1. 공유된 X 글에서 실제로 확인된 내용

    1-1. Gencoin8의 해석

    공유한 글은 “Astra를 사용하기 전에 AGENTS.md와 Skills를 정리하라”는 메시지와 함께, 과거에는 규칙·스킬·프롬프트를 계속 추가하는 방식이 유효했지만 이제는 “무엇을 더할까”보다 “무엇을 뺄까”가 중요해질 수 있다고 설명한다.[1]

    이 설명은 문제의식을 잘 잡았지만, 글 전체가 OpenAI의 공식 공지문은 아니다. 글에서 인용한 직접 근거는 Victor E. Nunez의 X 게시글이다.[1][2]

    1-2. Victor E. Nunez의 실제 발언

    Victor E. Nunez는 Astra rollout을 시작하면서 다음 세 가지를 다시 살펴볼 좋은 시점이라고 말했다.

  • AGENTS.md를 재검토하고 정리하기
  • Skills를 재검토하고 정리하기
  • reasoning level을 어떻게 사용할지 다시 생각하기
  • 또한 Astra Light가 빠르면서도 대부분의 작업에 충분히 능력 있다고 평가했다.[2]

    여기에는 “모든 스킬을 삭제하라”는 지시가 없다. 핵심은 모델이 바뀌면 기존 지침의 전제도 다시 검토하라는 것이다.

    1-3. Eric Provencher의 보충 설명

    OpenAI Codex 개발 경험팀의 Eric Provencher는 Skills, AGENTS.md, 작업 프롬프트가 지난 1년 동안 모델을 원하는 방향으로 유도하기 위해 점점 비대해졌을 수 있다고 설명했다.[3]

    그가 지적한 구체적인 문제는 다음과 같다.

  • Skill이 너무 많으면 이름·설명 목록이 길어져 선택에 필요한 정보가 흐려질 수 있다.
  • Skill 설명이 길거나 여러 Skill이 같은 작업을 주장하면 잘못된 Skill이 로드될 수 있다.
  • Skill 본문에 모든 절차를 넣기보다, 루트 SKILL.md는 필요한 자료를 가리키는 얇은 라우터로 두는 편이 낫다.
  • 모든 작업 전에 전체 문서·전체 저장소를 읽게 하는 AGENTS.md 규칙은 작은 작업에서 과도할 수 있다.
  • 작업의 “완료” 조건이 모호하면 Astra가 첫 번째 결과에서 멈추고 검토를 요청할 수 있으므로, 어디까지 하면 끝인지 프롬프트에 적어야 한다.[3]
  • 2. 공식 문서와 대조한 결과

    2-1. 공식 문서는 “감사하라”고 말한다

    OpenAI의 Astra 공식 API 가이드는 Astra가 이전 모델보다 일반적인 지시 이행 능력이 강하고, Skills나 AGENTS.md에 들어 있는 지시에 더 민감할 수 있다고 설명한다. 그래서 모델이 접근할 수 있는 Skills와 기타 파일을 감사하라고 강하게 권고한다.[4]

    즉, “지침이 많으면 무조건 나쁘다”가 아니라 지침의 영향력이 커졌으므로 오래된 지침과 충돌하는 지침을 방치하지 말라는 뜻으로 해석하는 것이 정확하다.

    2-2. Skill 자체는 여전히 유효하다

    OpenAI 공식 문서는 Skills를 반복 가능한 업무 흐름을 패키징하는 방식으로 설명한다. Skill은 지침·자료·스크립트를 묶어 특정 작업을 안정적으로 수행하게 하는 도구다.[6]

    다만 모델은 처음부터 모든 Skill 본문을 읽는 것이 아니라 이름과 설명을 먼저 보고 필요한 Skill을 선택한다. 따라서 설명은 짧고 범위가 분명해야 하며, 상세 자료는 필요할 때만 읽는 progressive disclosure 구조가 권장된다.[6]

    2-3. `AGENTS.md`는 없애는 파일이 아니라 계층적으로 관리하는 파일이다

    Codex는 전역·프로젝트·하위 디렉터리의 AGENTS.md를 계층적으로 읽으며, 더 가까운 위치의 지침이 뒤에서 우선한다.[5]

    따라서 AGENTS.md에는 모델이 추론해서 알기 어려운 다음 내용만 남기는 것이 좋다.

  • 프로젝트의 고유한 브랜드·독자·배포 규칙
  • 반드시 지켜야 할 보안·데이터·저작권 경계
  • 반복적으로 발생하는 실제 실수와 그 예방 규칙
  • 완료 판정에 필요한 프로젝트 고유 기준
  • 반대로 모든 작업에 적용되는 장황한 튜토리얼, 파일 전체를 읽으라는 습관성 지시, 이미 모델이 잘 수행하는 일반 행동은 우선 정리 대상이다.[3][5]

    2-4. Reasoning level은 높을수록 좋은 것이 아니다

    OpenAI의 Codex 모델 문서는 작업에 필요한 결과를 내는 가장 낮은 reasoning effort에서 시작하고, 계획·분석·검증이 더 필요한 작업일 때만 높이라고 안내한다.[7]

    권장 출발점은 다음과 같다.

  • Light / Low: 추출, 분류, 단순 변환, 반복 작업
  • Medium: 일반적인 작성·수정·조사 작업
  • High 이상: 여러 단계의 판단, 복잡한 코드, 상충하는 자료의 분석
  • Max / Ultra: 가장 어려운 단일 문제 또는 여러 하위 작업으로 나눌 수 있는 큰 작업
  • Astra Light가 빠르고 충분히 강하다는 Victor의 평가는 이 사용 패턴과 연결된다. 모든 작업을 최고 reasoning으로 돌리기보다, 작업별로 필요한 깊이를 선택하는 쪽이 대비책이다.[2][7]

    3. 과장과 사실을 분리해 보기

    사실에 가까운 주장

  • 모델이 더 강해질수록 오래된 지시가 예상보다 강하게 실행될 수 있다.[3][4]
  • Skills와 AGENTS.md에 충돌·중복·과잉 지시가 있으면 모델의 선택과 작업 흐름을 방해할 수 있다.[3][4]
  • Astra에서는 reasoning level과 작업 완료 기준을 다시 조정할 가치가 있다.[2][4][7]
  • 작업을 더 많이 맡길수록 실행 권한과 안전 경계를 명확히 해야 한다. OpenAI는 Astra를 중요한 사이버보안 능력의 임계 수준으로 평가했고, 일부 고급 능력은 제한적으로 제공한다고 설명했다.[8][9]
  • 그대로 믿으면 안 되는 주장

  • “Astra가 나오면서 기존 Skills가 전부 무용해졌다.”
  • “코딩 관련 Skills는 무조건 해롭다.”
  • “AGENTS.md를 전부 지워야 한다.”
  • “reasoning을 항상 낮춰야 한다.”
  • 공식 문서는 Skill과 AGENTS.md를 계속 유효한 확장 장치로 다루며, 좋은 지침은 오히려 모델의 행동을 더 예측 가능하게 만들 수 있다고 설명한다.[4][5][6]

    4. 디오 환경에 대한 현재 판정

    유지해도 되는 것

  • /Users/macmini/ai-creator-bus-site/AGENTS.md
  • - AI NOOK와 Workflow Radar의 독자 관점, 색상, 카드 구조, 발행 절차처럼 일반 모델이 알 수 없는 고유 규칙을 담고 있다.

    - 내용이 비교적 짧고, 브랜드·출력물의 품질 기준에 직접 연결된다.

  • /Users/macmini/dio-ai-talktalk-site/AGENTS.md
  • - AI 톡톡의 독자, 톤, 발행 일정, 배포 규칙을 담고 있다.

    - 역시 프로젝트 고유 정보이므로 삭제보다 중복 여부만 점검하는 것이 맞다.

  • ~/.agents/skills의 도메인별 Skills
  • - 현재 74개의 SKILL.md가 확인되지만, 개수가 많다는 이유만으로 전량 삭제하면 안 된다.

    - 각 Skill이 실제로 고유한 도구·API·안전 절차·반복 업무를 담는지 확인해야 한다.

    우선 점검할 것

  • 전역 ~/.codex/AGENTS.md는 현재 비어 있으므로, 이 파일 자체를 줄이는 작업은 필요 없다.
  • 프로젝트별 AGENTS.md에 “항상”, “모든 작업 전에”, “절대” 같은 전면 규칙이 더 추가되어 있는지 확인한다.
  • Skills의 description이 너무 넓어 관련 없는 작업에도 호출될 여지가 있는지 확인한다.
  • 여러 Skill이 같은 작업을 설명하거나 서로 다른 절차를 지시하는지 확인한다.
  • “사용자 승인 전에는 아무것도 하지 않는다”와 “작업 완료까지 자율적으로 진행한다”처럼 충돌하는 지침이 서로 다른 계층에 있는지 확인한다.
  • 5. Astra 전환 대비 실행안

    1단계 — 삭제하지 말고 기준선 만들기

    먼저 다음 네 종류를 목록으로 만든다.

    1. 전역 지침: ~/.codex/AGENTS.md

    2. 프로젝트 지침: 각 저장소의 AGENTS.md

    3. Skill 목록: 이름, description, 실제 사용 목적

    4. 작업 프롬프트: 반복해서 복사하는 긴 프롬프트와 템플릿

    각 항목에 다음 다섯 가지 태그 중 하나를 붙인다.

  • 고유 지식: 모델이 일반적으로 알 수 없는 정보
  • 안전 경계: 삭제하면 위험한 행동을 막는 규칙
  • 출력 계약: 결과물 형식과 완료 기준
  • 반복 절차: 특정 작업에서만 필요한 실행 방법
  • 구형 보정: 예전 모델의 부족함을 보완하려고 넣은 장황한 지시
  • 마지막 태그가 붙은 항목부터 검토한다. 바로 삭제하지 말고 원문을 보존한 채 후보로 표시한다.

    2단계 — Skill은 “얇은 라우터”로 줄이기

    좋은 Skill의 기본 형태는 다음과 같다.

    ---
    name: specific-workflow
    description: Use when doing one clearly defined workflow; not for adjacent tasks.
    ---
    
    # 목적
    이 Skill이 해결하는 한 가지 작업
    
    # 시작 조건
    언제 이 Skill을 읽어야 하는가
    
    # 완료 조건
    무엇이 되면 끝인가
    
    # 상세 자료
    필요할 때만 읽을 references/ 또는 실행할 scripts/
    

    정리 기준은 다음과 같다.

  • description에는 “무엇이든 관련되면 사용” 같은 넓은 표현을 쓰지 않는다.
  • Skill 하나가 너무 많은 업무를 떠안으면 분리하거나 라우터와 상세 자료를 나눈다.
  • 다른 Skill과 같은 트리거를 쓰면 범위를 좁힌다.
  • 모델이 이미 자연스럽게 판단하는 일반 행동은 반복해서 강제하지 않는다.
  • 반대로 프로젝트 고유 API, 브랜드 기준, 보안 절차, 실패하기 쉬운 명령은 남긴다.
  • 3단계 — `AGENTS.md`는 예외와 기준 중심으로 다시 쓴다

    다음과 같은 문장은 줄일 후보이다.

    모든 작업 전에 저장소 전체를 읽고 전체 구조를 파악한다.
    모든 변경 후 전체 테스트를 실행한다.
    어떤 작업이든 다음 단계로 가기 전에 매번 승인을 요청한다.
    

    다음처럼 범위와 완료 기준을 붙이는 편이 낫다.

    인증·배포·결제·삭제처럼 되돌리기 어렵거나 외부 시스템에 영향을 주는 작업은 실행 전에 확인한다.
    로컬 파일 수정과 읽기 전용 조사처럼 되돌릴 수 있는 작업은 요청한 범위 안에서 진행한다.
    작업 완료는 결과 파일 생성, 필요한 검증, 핵심 결과 보고까지로 본다.
    

    핵심은 안전 경계를 지우는 것이 아니라, 사소한 작업까지 막는 전면 규칙과 실제 위험한 작업을 구분하는 것이다.

    4단계 — reasoning과 완료 기준을 작업별로 조정한다

    작업 프롬프트에 아래 두 줄을 기본으로 넣는다.

    이 작업의 완료 조건은 다음과 같다: [결과물]을 만들고, [검증]을 수행한 뒤, [보고 내용]까지 남긴다.
    작업을 중간 결과에서 멈추지 말고 위 완료 조건을 만족할 때까지 진행하되, 되돌릴 수 없거나 외부 시스템에 영향을 주는 작업은 실행 직전에 확인한다.
    

    그 뒤 작업 성격에 따라 reasoning을 선택한다.

  • 자료 정리·변환: Light/Low
  • 일반 콘텐츠 작성·리서치·로컬 수정: Medium
  • 복잡한 설계·코드·여러 자료의 충돌 분석: High 이상
  • 높은 reasoning을 기본값으로 고정하지 말고, 결과 품질·시간·사용량을 실제 작업으로 비교한다.

    5단계 — 작은 A/B 테스트로 판단하기

    전환 전에 다음 세 작업을 기존 설정과 Astra에서 각각 한 번씩 실행한다.

    1. 짧은 문서 수정

    2. 여러 파일을 읽고 요약하는 작업

    3. 로컬 프로젝트의 작은 기능 수정과 검증

    아래를 기록한다.

  • 첫 결과까지 걸린 시간
  • 불필요한 파일 읽기와 테스트가 있었는지
  • 중간에 불필요하게 멈추거나 승인을 요청했는지
  • 지침 충돌이나 잘못된 Skill 호출이 있었는지
  • 최종 결과의 품질과 수정 횟수
  • 사용량 또는 비용
  • Astra가 잘한 작업만 보고 전환하지 말고, 기존 지침이 방해한 사례를 찾는 것이 목적이다.

    6. 디오에게 맞는 실전 원칙

    1. 지금 당장 Skills를 지우지 않는다. 먼저 목록화하고 3개 작업으로 검증한다.

    2. 브랜드·배포·보안처럼 모델이 알 수 없는 규칙은 남긴다. AI NOOK와 AI 톡톡의 프로젝트 헌법은 현재 역할이 분명하다.

    3. 고유 지식은 Skill에 남기고, 작업마다 필요한 순서는 프롬프트나 references로 분리한다.

    4. 읽기·분석·초안 작성은 자율성을 높이고, 배포·외부 게시·삭제·결제·권한 변경은 사람 확인을 유지한다. Astra의 능력이 커져도 실행 권한의 경계까지 자동으로 넓혀서는 안 된다.[8][9]

    5. “더 자세히 지시하기”보다 “무엇이 끝인지 명확히 말하기”를 우선한다.

    6. 모델을 바꿀 때마다 규칙을 다시 평가한다. 한 번 정리하고 영구 고정하는 것이 아니라, 다음 모델 업데이트 때 다시 작은 회고를 한다.

    7. 바로 사용할 감사 프롬프트

    이 프로젝트를 GPT-6 Astra에 맞게 감사해줘.
    
    목표는 파일을 무작정 삭제하는 것이 아니라, 현재 지침이 작업을 돕는지 방해하는지 판별하는 것이다.
    
    검사 대상:
    1. AGENTS.md와 하위 지침 파일
    2. 설치된 Skills의 name과 description
    3. 반복해서 사용하는 긴 작업 프롬프트
    
    각 항목을 다음 중 하나로 분류해줘:
    - 유지: 고유 지식·안전 경계·출력 계약에 필요
    - 축약: 내용은 필요하지만 문장이 과도함
    - 분리: 항상 읽히는 내용과 특정 작업용 내용을 나눠야 함
    - 통합: 다른 지침과 중복됨
    - 보류: 실제 작업 사례를 더 본 뒤 결정
    
    각 판단에는 다음을 포함해줘:
    - 정확한 파일 경로
    - 문제가 되는 문장 또는 description
    - 왜 Astra에서 방해가 될 수 있는지
    - 삭제하지 않고 안전하게 고치는 제안
    
    절대 파일을 수정하지 말고, 먼저 감사 보고서만 작성해줘.
    

    최종 판단

    Astra는 “프롬프트를 더 많이 써야 하는 시대”의 끝이라기보다, 모델에게 맡길 판단과 사람이 직접 고정해야 할 경계를 다시 나누는 계기에 가깝다.

    디오에게 필요한 대비는 다음 한 문장으로 정리된다.

    **스킬 수를 줄이는 것이 목표가 아니라, 모델이 몰라도 되는 절차는 빼고 모델이 알 수 없는 지식과 안전 경계만 남기는 것.**

    관련 노트

  • [[AI 파트너 진단 질문지]]
  • [[Cloudflare Pages 배포 방식 비교]]
  • [[Anthropic Cybersecurity Skills 방어형 10개 Hermes 설치 및 사용법]]
  • 지식 후보 판단

    knowledge-candidate: true

    모델 세대가 바뀔 때마다 AGENTS.md·Skills·프롬프트를 감사하는 재사용 가능한 운영 원칙과 체크리스트를 담고 있어, 이후 Hermes·Codex·Claude Code 운영 문서로 확장할 가치가 있다.

    Sources

    [1] https://x.com/gencoin8/status/2096107750589857989?s=46 — Gencoin8의 Astra 관련 X 게시글

    [2] https://x.com/victornunez/status/2095895077381972247 — Victor E. Nunez의 Astra rollout 관련 X 게시글

    [3] https://x.com/pvncher/status/2095991462416490862 — Eric Provencher의 GPT-6 Astra Skills/프롬프트 재검토 글

    [4] https://developers.openai.com/api/docs/guides/latest-model — OpenAI API Model guidance: GPT-6 Astra

    [5] https://developers.openai.com/codex/agent-configuration/agents-md — OpenAI Codex AGENTS.md 공식 문서

    [6] https://developers.openai.com/codex/build-skills — OpenAI Codex Build skills 공식 문서

    [7] https://developers.openai.com/codex/models — OpenAI Codex Models 공식 문서

    [8] https://openai.com/index/path-to-astra — OpenAI Path to Astra: safeguards

    [9] https://www.axios.com/2026/09/03/openai-astra-gpt-6-agi-brockman — Axios: OpenAI releases GPT-6 Astra